Richard Sutton
Apparence
Richard S. Sutton
Naissance | |
---|---|
Nationalité | |
Domicile | |
Formation | |
Activités |
A travaillé pour | |
---|---|
Membre de | |
Directeur de thèse |
Andrew Barto (en) |
Distinction |
Richard Sutton est un informaticien canadien, enseignant en informatique à l'université de l'Alberta. Il est considéré comme l'un des fondateurs de l'apprentissage par renforcement, domaine auquel il a apporté plusieurs contributions majeures telles que le temporal difference learning et les méthodes de gradient.
Formation
[modifier | modifier le code]Sutton a reçu son B.A. en psychologie à l'université Stanford en 1978, et ses M.Sc. et Ph.D en informatique à l'université du Massachusetts à Amherst en 1980 et 1984, sous la direction d'Andrew Barto (en). Sa thèse, « Temporal Credit Assignment in Reinforcement Learning », introduisait en particulier des idées de temporal difference learning.
Publications
[modifier | modifier le code]- (en) Sutton, R. S., Barto, A. G., Reinforcement Learning: An Introduction. MIT Press, 1998. 2e édition MIT Press en 2018.
- (en) Miller, W. T., Sutton, R. S., Werbos, P. J. (Eds.), Neural Networks for Control. MIT Press, 1991.
- (en) Sutton, R. S. (Ed.), Reinforcement Learning. Reprinting of a special issue of Machine Learning Journal. Kluwer Academic Press, 1992
Références
[modifier | modifier le code]- (en) Cet article est partiellement ou en totalité issu de l’article de Wikipédia en anglais intitulé « Richard S. Sutton » (voir la liste des auteurs).
- (en) Richard Sutton, « Brief Biography for Richard Sutton » (consulté le )
- (en) « University of Massachusetts Amherst School of Computer Science Outstanding Achievement and Advocacy Award - 2013 » (consulté le )
Liens externes
[modifier | modifier le code]
- Ressources relatives à la recherche :